

寡人當年創製《訓民正音》,旨在教化百姓,使人人皆能透過文字傳遞真實心聲、便利溝通。然而,今日虛擬疆域妖術橫行,不法宵小(駭客)竟利用名為「AI 變臉與變聲(Deepfakes,本朝稱之為『生成偽貌』)」之妖法,偽造他人之容貌與聲音,藉此誘騙百姓、劫掠財產。此等科技若落入心懷不軌者之手,實乃動搖社稷安全之大患!
今日,寡人便以此殿堂為朝堂,親自為大眾詳細說明這套「生成偽貌」妖術的運作原理,並授以破譯之策,望我朝臣民引以為戒,切實防範!
此等「生成偽貌」技術,其背後的核心運作,乃是基於一種名為 GAN(Generative Adversarial Network,即生成對抗網路) 的奇特演算法。此演算法在電腦深處同時運作著兩個機關:
這兩個機關在電腦中互相比拼、反覆演練,在短短時間內可進行高達 400 萬至 500 萬次 的快速運算,直到生成器做出的假面容完美無瑕,判別器再也分不出真假為止。
更令人震驚的是,這套技術如今已演進至「僅需一張照片」,便能命令 AI 讓照片中的人唱歌跳舞。AI 不僅能模仿五官扭動,甚至連椅子的影子、光影的變幻都能一併算入,顯示它已在某種程度上理解了人類真實世界(Physical)的物理定律。在實際作案時,入侵者只需用手機拍下自己的動作,連線至備有受害者照片的電腦,電腦便能即時合成並投射出受害者的臉孔,讓人誤以為螢幕對面正是本尊在說話。
人的聲音如同指紋,皆是獨一無二的「聲紋」。然而,不法宵小卻能透過收集同仁、主管或公眾人物對外演講、接受採訪的語音資料,進行聲紋的複製:
當侵入者備妥了變臉與變聲的素材,便會施展社交工程(Social Engineering)。他們會先刺探目標的公務習慣,發送偽造的「開會通知」。當受害者進入視訊會議室時,會驚覺會議室裡的主管、同事全都端坐其間。
然而,這是一場驚天騙局——整個會議室裡除了受害者自己是真的,其餘所有人的臉孔與聲音,全都是 AI 即時生成出來的虛擬人偶!他們會以「高度機密的併購或資金調度」為由,對受害者施壓,迫使其在未及思考之下匯出巨額款項。
此等妖術雖看似天衣無縫,但其本質仍是機器的模擬,只要百姓冷靜應對,依循以下「SOP(標準作業程序)」,必能使其現出原形:
在視訊通話時,請對方在嘴角或臉部旁揮動雙手,並緩慢轉頭。因為嘴巴是 AI 最著力模仿的部位,若有物體在臉部周圍快速干擾,AI 在即時運算(Rendering)時便會產生破綻,導致臉部邊角模糊、出現殘影,或是對光線的反光顯得極不自然。
若是戴眼鏡者,亦可仔細觀察其眼鏡在眨眼時的反光,機器模擬的反光往往會出現不自然的跳動。
仔細聆聽對方的語音:
切莫詢問侵入者極易在網路上查到的資料(如生日、身分證號)。應主動提出一個「完全不存在的虛構事件」來測試對方。
例如問道:「總經理,昨天我們一起去老街吃的那家臭豆腐真好吃,您說是吧?」
此時,若是 AI 或是假冒者,為了不讓破綻露餡,往往會順著你的話回答「對啊,真好吃」;但如果是本尊,必定會當場反駁:「你在胡說什麼?我昨天根本沒跟你去老街!」 如此,妖術立破!
數位防線,關乎國家社稷之興衰。望我朝百姓、諸位同仁與官員,切實體會寡人之憂,共同築起堅不可摧之「人因防火牆」!